扫描下载APP
其它方式登录
OpenAI推出GPT-Live实时语音模型,采用全双工架构实现边听边说,并与GPT-5.5协同完成搜索、推理等复杂任务,使ChatGPT语音交互在架构上追平豆包Seeduplex和Gemini Live;三者虽均支持全双工,但技术侧重不同:豆包强于中文口语识别与抗干扰,Gemini强调多模态实时感知,GPT-Live聚焦语音中深度思考与任务执行。
OpenAI发布新一代语音模型GPT-Live,采用全双工(full-duplex)架构,实现边听边说、实时响应、短反馈等自然对话能力,驱动ChatGPT Voice升级;虽技术进步显著,但用户反馈两极分化,部分人认为其频繁插话和短反馈令人烦躁,且暂不支持语音/视频通话及屏幕共享功能。
OpenAI发布全新语音模型GPT-Live,采用全双工架构实现边听边说,支持自然对话交互(如垫话、静默等待、抗干扰),并解耦前台交互与后台推理(调用GPT-5.5等前沿模型),显著提升流畅度、推理准确率与Agent能力,标志着语音从功能升级为统领多模态的超级入口。